一起来看一下成品:
准备工具
flowpix https://www.flowpix.club/
https://www.flowpix.club/bj/40058.html?token=72b05b7308ac3b82cce74aacbef7368a
第一步:把产品图片上传到 FlowPix
打开 FlowPix,新建一个画布。
把准备好的产品图片全部上传到画布中。
这次我准备了三张不同类型的素材:
小米 SU7 内饰图

用来测试汽车内饰类宣传视频。
iPhone 17 Pro Max 产品图

用来测试数码产品类宣传视频。
迈从键盘产品图

用来测试桌面外设类宣传视频。
这里不需要提前制作复杂的分镜,也不需要自己写 MiniMax H3 提示词。
我们只需要准备几张能够清楚展示产品特征的图片。
第二步:让 Agent 帮我们设计视频
图片上传完成后,打开 FlowPix 中的 Agent。

模型选择:
Kimi K3

然后在画布中选择需要制作视频的产品图片。

这里先以小米 SU7 的内饰为例。
我第一次直接告诉 Agent:
“这是小米SU7的内饰,我想用AI做一个汽车内饰宣传视频,我会使用minimax h3的模型去生成视频。我需要提示词,符合minimax h3的提示词要求,要展现出内饰的年轻活力与运动感。帮我想一下视频提示词。”

Agent 会根据图片识别产品,并开始生成对应的视频提示词。
也就是说,我们真正需要告诉 AI 的并不是复杂的运镜、景别、节奏和光影参数。
只需要说清楚:
这是什么产品 + 想做什么视频 + 想要什么感觉。
剩下的镜头设计可以先交给 Agent。

第三步:调整Agent提示词
第一次生成之后,我发现还有一个问题。
Agent 虽然能够写提示词,但它并不一定完全理解我们接下来使用 MiniMax H3 的具体生成方式。
如果不进一步说明,它很容易把上传的参考图理解成:
尽量保持原来的画面和构图,再让画面发生运动。
但这并不是我想要的结果。
我希望产品本身保持一致,但镜头可以重新设计。
所以我继续告诉 Agent:
“只需要给我视频提示词,我用的是全能参考模式。”

这句话非常重要。
它相当于告诉 Agent:
参考图片主要负责提供产品信息,而最终的视频镜头可以拥有更大的设计空间。
接下来我又增加了一条要求:
“我给的图片仅做内饰参考,不要完全使用我所给图片的镜头,镜头需要你自己设计,符合高端TVC审美。”

这一句主要解决一个非常常见的问题:
参考图是什么构图,AI 就一直围绕这个构图生成。
比如原图只是一个普通的汽车内饰正面照片。
如果直接图生视频,最终很可能只是:
镜头轻微推进、灯光变化、方向盘稍微运动。
产品虽然动起来了,但并没有真正形成一支广告片。
例如这样
反面案例
而加入这条要求后,我们实际上是在告诉 Agent:
保留产品,而不是保留照片。产品的材质、造型和设计语言来自参考图。但是:景别可以重新设计。机位可以改变。运镜可以重新安排。灯光可以变化。产品局部可以被重新展示。
这样生成出来的提示词,才更接近真正的视频分镜,而不是单纯让一张产品图动起来。
等 Agent 生成完整的视频提示词以后,接下来就非常简单了。
在 FlowPix 中:
框选你的图片,拉出一条线,选择生成视频,随后选择Mini MAX h3

然后把 Agent 刚刚生成的视频提示词直接放进去。
提示词如下:
图像1、图像2、图像3、图像4仅作为小米SU7砂陶米内饰的材质与配色参考:米白色 打孔皮革、菱形绗缝工艺、冰蓝色氛围灯、悬浮式中控屏、全景天窗,视频中的内饰 质感须与参考图一致,但镜头角度与构图不限于参考图。 一段高端汽车内饰TVC:黑场中一束光扫过米白色打孔皮革座椅表面,皮革纹理与 菱形绗缝在侧光中渐次浮现;镜头沿座椅缝线极速滑行,转场至冰蓝色氛围灯在 暗部沿门板流动的光轨;低角度仰拍,方向盘红色装饰按键在光影中掠过,中控 大屏从黑暗中点亮,冷光映在皮革上;镜头穿过中央扶手区向上摇升,全景天窗 外天光倾泻而下,整个座舱在晨曦中苏醒;最终镜头从车顶俯瞰角度环绕座舱一 周,在对称构图的座舱全景中缓缓定格。全程运用微距质感镜头、光影对比、 速度感运镜与呼吸感节奏,暗调与高光交替,质感冷峻高级,充满年轻活力与 运动张力,国际一线汽车广告制作水准,电影级调色。
最后点击生成即可。
到这里,一条产品宣传视频就完成了。
第四步:换一个产品,不需要重新研究提示词
这个方法比较方便的一点,是它不局限于汽车。
比如接下来我要制作 iPhone 的产品宣传视频。
只需要把 iPhone 图片加入 Agent,然后直接告诉它:
这是iphone 17promax 同样的仅作参考生成15s tvc宣传视频。主要宣传手机的镜头。帮我想一下视频提示词】

Agent 就会重新根据手机这个产品设计视频提示词。
视频提示词如下:
图像1、图像2、图像3仅作为iPhone 17 Pro Max星宇橙配色的材质参考:橙色金属中框、磨砂玻璃背板、横向圆角矩形三摄模组、黑色镜头玻璃与闪光灯开孔,视频中的机身质感与配色须与参考图一致,但镜头角度与构图不限于参考图。
一段15秒高端手机TVC,主角是摄像头:黑场中一道冷光缓缓扫过镜头玻璃表面,镀膜反射出深邃的蓝紫色光泽;微距镜头推进,三颗镜头如精密仪器般从暗影中浮现,镜头边缘的金属倒角闪过一道高光;镜头极速环绕相机模组一周,橙色金属机身在光影流动中显现,磨砂背板与亮面中框形成材质碰撞;视角穿越镜头玻璃进入光学结构内部,镜片组层层展开、光路在镜筒中折射穿行;镜头拉出,手机在深色空间中缓缓旋转升起,一束顶光打亮整个相机模组;最终手机定格于画面中央,镜头模组朝向观众,反射出一点星芒。全程运用微距质感镜头、明暗对比、速度感环绕运镜与呼吸感节奏,冷峻高级,充满科技精密感与力量感,国际一线科技广告制作水准,电影级调色。
接下来依然是:
Agent 生成提示词 → 创建 MiniMax H3 节点 → 连接产品图 → 生成视频。
换成键盘也是一样。
告诉 Agent:
前4张图片是这款键盘的轴体爆炸图以及键盘爆炸图,后面3张是三款不同的键盘颜色,同样的仅作参考生成15s tvc宣传视频。需要展现三款颜色(丝滑变换),以及展现键盘轴体,还有键盘本身。帮我想一下视频提示词

它就会围绕键盘重新设计镜头。
所以这里真正可以复用的,不是一条固定的视频提示词,而是生成提示词的方法。
最后
以前使用 AI 做产品视频,我们很容易把大量时间花在“怎么写提示词”上。
但当 Agent 和视频模型结合以后,流程可以发生变化。
产品图片负责告诉 AI“拍什么”。
我们负责告诉 Agent“想拍成什么感觉”。
Agent 负责设计镜头和提示词。
MiniMax H3 负责把它真正生成出来。
这样一来,换汽车、手机、键盘,甚至换成其他产品,都不需要从头学习一套新的提示词。
对于日常产品视频制作来说,这种方式真正提升的不是某一条视频的效果,而是整个产品视频的制作效率。
视频生成执行卡
把这节课压缩成一张可执行卡片:看重点、照步骤、避坑,再复制模板直接开做。
这节课不是先追求炫技成片,而是围绕「刺猬星球super-i_AI教程免费在线教学」先把主体、动作、镜头和节奏稳住。
按原文节奏走最稳:先吃透「准备工具」,再把「第一步:把产品图片上传到 FlowPix」定住,接着处理「第二步:让 Agent 帮我们设计视频」;最后用「第三步:调整Agent提示词」收口。
- 先把「准备工具」里的主体和动作定死。
- 这一段重点看镜头和节奏,别急着炫技。
- 做完「第二步:让 Agent 帮我们设计视频」后,先查连贯性和穿帮。
- 把「第三步:调整Agent提示词」整理成可复制版本,后面直接复用。
- 把「第四步:换一个产品,不需要重新研究提示词」整理成可复制版本,后面直接复用。
- 做完「最后」后,先查连贯性和穿帮。
不要一上来就生成最终片;先拆镜头、定主体和运动,再逐段生成,否则容易跳轴、穿帮、节奏混乱。
检查主体是否稳定;镜头运动是否明确;前后画面是否连贯;节奏是否服务主题;是否有明显变形或穿帮。
请围绕「刺猬星球super-i_AI教程免费在线教学」帮我做一个可直接执行的方案。 我的目标是:【填写你的具体目标】 我的素材/产品/角色信息是:【填写已有素材和限制】 请输出:核心创意、分镜表、每个镜头的画面描述、视频生成提示词、剪辑顺序和成片自检清单。要求主体稳定、动作明确、镜头连贯。